新一代具身推理模型Gemini Robotics ER2發佈,專爲硬件打造,顯著提升物理環境理解與多步驟任務規劃能力,並首次攻克多機器人協同作業難題,加速人形機器人落地迭代。
Google DeepMind發佈新一代音樂生成模型Lyria3.5,在音樂性、歌詞與人聲表現力及創作控制上大幅提升,可構建更復雜自然的旋律織體,推動AI音樂向專業應用邁進。
谷歌DeepMind已悄然解散曾獲諾貝爾化學獎的AlphaFold團隊。該系統的核心人物哈薩比斯與江珀剛在2024年憑此獲獎,但過去一年中,多數原始論文作者已被重新分配至其他項目,這支明星團隊正被悄然拆解。
谷歌DeepMind因員工士氣低迷推遲發佈Gemini 3.5 Pro,模型已落後原計劃數月。近期推出的小模型市場反應褒貶不一,遭Meta AI負責人汪滔公開嘲諷。團隊正經歷嚴重人才流失,軍方合約被指加劇離心,Gemini聯合負責人諾姆·沙澤爾亦被曝離職。
Veo 4 是 Google DeepMind 的 AI 視頻生成與圖像編輯平臺。
Google DeepMind旗艦多模態AI,1M上下文,具備博士級推理與高級編碼能力
Nano Banana 2 是由 Google DeepMind 開發的專業 AI 圖像編輯器。
Google DeepMind推出的最先進的AI天氣預報技術。
Google
-
輸入tokens/百萬
輸出tokens/百萬
上下文長度
$0.14
$0.28
131
$1
$17.5
$70
2.1k
brittlewis12
Gemma 3 4B IT GGUF 是 Google DeepMind 推出的輕量級開源語言模型,基於與 Gemini 模型相同的研究和技術構建。該模型具有 128K 的大上下文窗口,支持超過 140 種語言,採用 GGUF 格式便於在各種設備上部署運行。
Gemma 3 1B IT GGUF 是 Google DeepMind 開發的輕量級開源語言模型的 GGUF 格式版本。該模型基於 Gemma 3 1B IT(指令微調)模型轉換而來,具有 128K 的大上下文窗口,支持超過 140 種語言,適合在資源有限的環境中部署。
Crystalcareai
GemMoE 是基於 Deepmind 的 Gemma 架構的專家混合(MoE)模型,融合了 8 個單獨微調的 Gemma 模型,每個令牌配備 2 個專家,功能強大且易於訓練和推理。
HuggingFaceM4
IDEFICS是Deepmind開發的閉源視覺語言模型Flamingo的開源復現版本,支持多模態輸入(圖像+文本)並生成文本輸出。
IDEFICS 是 Deepmind 開發的閉源視覺語言模型 Flamingo 的開源復現版本,是一個多模態模型,可以接受任意序列的圖像和文本輸入,並生成文本輸出。
IDEFICS是一個開源的多模態模型,能夠處理圖像和文本輸入並生成文本輸出,是Deepmind Flamingo模型的開源復現版本。
IDEFICS-9B是一個90億參數的多模態模型,能夠處理圖像和文本輸入並生成文本輸出,是Deepmind Flamingo模型的開源復現版本。
deepmind
Perceiver IO是一種通用Transformer架構,可處理多種模態數據,本模型專為圖像分類任務設計,在ImageNet數據集上預訓練。
基於ImageNet預訓練的通用視覺感知器模型,採用卷積預處理和Transformer架構,支持圖像分類任務
oandreae
該模型是基於deepmind/language-perceiver在financial_phrasebank數據集上微調的金融文本情感分類模型。
基於BERT的掩碼語言建模任務預訓練,支持處理UTF-8字節輸入的多模態Transformer模型
基於ImageNet預訓練的通用視覺感知器模型,採用學習型位置嵌入處理圖像輸入